Управление на европроекти управление на европроекти
Claude

Anthropic обвинява DeepSeek и други китайски AI лаборатории в злоупотреба с Claude чрез „дистилация“

Anthropic заяви, че три големи AI лаборатории от Китай — DeepSeek, MiniMax и Moonshot AI — са използвали Claude „незаконно“, за да ускорят развитието на собствените си модели. Според компанията става дума за мащабни операции, които заобикалят ограниченията за достъп и нарушават условията за ползване.

Anthropic добавя, че подобни практики стават все по-интензивни и по-сложни и изискват бързи, координирани действия от индустрията, регулаторите и глобалната AI общност.

Какво твърди Anthropic за DeepSeek, MiniMax и Moonshot AI

По данни на Anthropic трите лаборатории са използвали процес, известен като „дистилация“, за да извличат способности от Claude и да ги пренасят в по-слаби или по-евтини модели. Компанията описва тези усилия като „индустриални“ кампании, включващи приблизително 24 000 фалшиви акаунта в Claude и над 16 милиона обмена (запитвания и отговори), извършени в нарушение на условията за ползване и регионалните ограничения за достъп.

Anthropic посочва, че Claude не е достъпен за търговска употреба в Китай, но според компанията конкурентите са намирали начини да заобиколят това ограничение.

Как работи „дистилацията“ и защо е спорна

„Дистилацията“ представлява обучение на по-малък или по-малко мощен модел върху изхода (отговорите) на по-силен модел. Самият метод може да бъде легитимен и се използва от редица компании в САЩ, включително за подготовка на модели за публично пускане. В последно време обаче големи американски компании все по-често твърдят, че китайски конкуренти прилагат дистилация неправомерно, за да „копират“ способности и да съкратят времето и разходите за разработка.

-25% ОТСТЪПКА ОТ ХОСТИНГ jump.bg намаление
Anthropic предупреждава, че неправомерната дистилация може да доведе до модели с по-слаби защити и по-високи рискове, включително при злоупотреби, свързани с опасни биологични приложения.

Детайли за предполагаемите кампании и реакциите в сектора

Сред примерите, цитирани от Anthropic, е твърдение, че DeepSeek е търсила начини да създава „алтернативи, устойчиви на цензура“ при запитвания, чувствителни от гледна точка на политики. Компанията също така заявява, че е засекла кампанията на MiniMax, докато тя още е била активна, което е дало възможност за по-детайлен поглед върху методите на конкурента.

Anthropic твърди, че при пускането на нов модел по време на активната кампания на MiniMax, лабораторията е променила поведението си в рамките на 24 часа и е пренасочила почти половината от трафика си, за да „улови“ способности от най-новата система.

В по-широк контекст Anthropic отбелязва, че и други компании съобщават за подобни сигнали: OpenAI заяви, че DeepSeek може да е използвала по неподходящ начин изходи на OpenAI за обучение, а Google оповести, че е идентифицирала ръст на опити за извличане на модели, описвани и като „дистилационни атаки“.

Мерки за защита, експортен контрол и спорни практики при данни

Anthropic съобщава, че в отговор е внедрила системи за „поведенческо профилиране“ (behavioral fingerprinting), споделя индикатори с други AI компании и разработва допълнителни контрамерки. Компанията аргументира, че подобни атаки засилват логиката за експортен контрол: ограниченият достъп до чипове би намалил както възможностите за директно обучение на модели, така и мащаба на неправомерната дистилация.

Позицията за експортните ограничения е предмет на разногласия сред технологичните лидери. Jensen Huang, главен изпълнителен директор на Nvidia, многократно е заявявал, че ограничаването на продажбите на усъвършенствани чипове от американски компании за Китай няма да спре напредъка на китайската AI индустрия.

Отделно от тези обвинения, Anthropic е обект и на критики относно използване на защитени с авторски права материали за обучение. Компанията постигна споразумение по колективен иск от автори и издатели за 1,5 млрд. долара, без да признава вина. Появиха се и сведения за вътрешна инициатива, наречена Project Panama, описвана като усилие за мащабно сканиране на книги.

Какво означава това

  • Ескалация на конфликта около „дистилацията“: практиката остава легитимен инструмент, но спорът се измества към това кога е неправомерно извличане на способности.
  • Повече инвестиции в защита: „поведенчески отпечатъци“, засичане на аномалии и споделяне на сигнали между компании вероятно ще станат стандарт.
  • Рискове за сигурността: ако по-слабо обучени модели наследят „умения“ без същите предпазни механизми, се увеличава рискът от опасни приложения.
  • Геополитически ефект: темата може да подкрепи аргументи за експортни контроли и по-строги ограничения за достъп до водещи AI модели.
  • Двойни стандарти и правни спорове: паралелно с обвиненията към конкуренти, продължават дебатите за това какви данни е допустимо да се използват за обучение.

Back to top button